A multiregional image-text dataset and benchmark for vision-language modeling of plant diseases
本論文は、多様な世界の作物システムにわたる255,000以上の画像・テキストペアからなるLeafNet 2.0データセットと、現実的な圃場条件下での微細な植物病害の検出および推論のための視覚言語モデリングを前進させるよう設計されたLeafBench 2.0ベンチマークからなる包括的なマルチモーダルリソースであるLeafMDを紹介するものである。